Skip to content
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit überlangen Kontexten gestaffelte Preise.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe berechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag von AI-ROUTER noch eine fehlerhafte Abrechnung dar.</p><p></p><p>Beispiel anhand der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgang $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und weiterer Abrechnungseinstellungen berechnet.</p><p></p><p>Wenn in den Nutzungsdaten das Kennzeichen x2 erscheint, bedeutet dies, dass für diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst wurde. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass alle Kosten der gesamten Anfrage einfach verdoppelt werden; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn Sie kein Kontextfenster von 1M Tokens benötigen, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprünglich im Artikel beschriebene 1M-Konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>in:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - sehr lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge umfangreicher Tool-Ausgaben in einer einzelnen Antwort zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn Sie tatsächlich ein Kontextfenster von 1M Tokens benötigen, können Sie die ursprüngliche Konfiguration weiterhin verwenden. Für den Anteil über 272K werden dann jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Die ursprüngliche Konfigurationsanleitung finden Sie hier: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie ein Kontextfenster von 1 Million Tokens für GPT-5.6 Sol in Codex </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>
  • 0 Votes
    1 Posts
    96 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit extrem langen Kontexten eine gestaffelte Preisstruktur.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe abgerechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag noch eine fehlerhafte Abrechnung durch AI-ROUTER dar.</p><p></p><p>Am Beispiel der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgänge $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und anderer Abrechnungseinstellungen berechnet.</p><p></p><p>Das x2-Kennzeichen in den Nutzungsdaten bedeutet, dass diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst hat. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass sich alle Kosten der gesamten Anfrage einfach verdoppeln; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn kein Kontextfenster mit 1M Tokens benötigt wird, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprüngliche Konfiguration für 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zu:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - besonders lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge der auf einmal zurückgegebenen Tool-Ausgaben zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn tatsächlich ein Kontextfenster mit 1M Tokens benötigt wird, kann die ursprüngliche Konfiguration weiterhin verwendet werden. Nach Überschreiten von 272K werden jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Eine Beschreibung der ursprünglichen Konfiguration finden Sie unter: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie in Codex ein Kontextfenster mit 1 Million Tokens für GPT-5.6 Sol </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>